AI资讯新闻榜单内容搜索-DeepSeek

笑不活了，“日本最高性能AI模型”，是DeepSeek V3改了个名？

3月17日，楽天（乐天）集团正式发布了Rakuten AI 3.0模型，号称是“日本国内最大规模的高性能AI模型”。官方宣传的参数量为约7000亿，并且日语特化，Apache 2.0开源许可，还拿了日本经产省和NEDO的GENIAC项目补助。

来自主题: AI资讯

8857 点击 2026-03-17 23:46

独家｜梁文锋将携DeepSeek V4撞上姚顺雨

我们独家获悉，外界千呼万唤的DeepSeek-V4将于4月正式上线。作为梁文锋打磨已久的多模态大模型，DeepSeek-V4除了在Coding能力上跃升之外，还将在LTM（long term memory长期记忆）上取得突破。

来自主题: AI资讯

11242 点击 2026-03-12 17:20

ICLR 2026｜早于DeepSeek Engram，STEM已重构Transformer「记忆」

近年来，随着大语言模型规模与知识密度不断提升，研究者开始重新思考一个更本质的问题：模型中的参数应如何被组织，才能更高效地充当「记忆」。

来自主题: AI技术研报

8694 点击 2026-03-10 09:31

OpenAI测谎13款大模型：Claude 3.7封神，GPT-5.2近乎失控！

OpenAI的最新研究揭示了一个反直觉的真相：越强大的推理模型，越管不住自己的「脑子」。在CoT-Control套件测试的13款前沿模型中，DeepSeek R1控制自身思维链的成功率仅为0.1%，Claude Sonnet 4.5也只有2.7%。

来自主题: AI资讯

9525 点击 2026-03-09 15:08

DeepSeek V4下周登场，美股再次颤抖！「跳过」英伟达，便宜50倍

DeepSeek V4下周登场：原生多模态，绕过英伟达，针对国产芯片深度优化。华尔街最怕的那条逻辑可能又要重演：算力霸权松动，美股先颤抖。

来自主题: AI资讯

9444 点击 2026-03-01 16:38

春节AI大战退潮，Claude被封杀Anthropic「单挑」中美，全民养「龙虾」｜Hunt Good 周报

所有人都在等 DeepSeek，春节来，下周来，还是没来。一场为了全面「狙击」 DeepSeek，抢夺流量，但是 DeepSeek 都没出现的春节大战，就在一轮又一轮的红包奶茶里轰轰烈烈地结束了。

来自主题: AI资讯

9160 点击 2026-03-01 10:56

DeepSeek新论文来了！联手清华、北大，优化智能体大模型推理

「DeepSeek V4 来了！」这样的消息是不是已经听烦了？总结来说，这篇新论文介绍了一个名为「DualPath」的创新推理系统，专门针对智能体工作负载下的大语言模型（LLM）推理性能进行优化。具体来讲，通过引入「双路径 KV-Cache 加载」机制，解决了在预填充 - 解码（PD）分离架构下，KV-Cache 读取负载不平衡的问题。

来自主题: AI技术研报

9158 点击 2026-02-27 11:35